Articles dans le thème: apprentissage automatique
Page 2
Gemma 4 : modèles MoE ouverts de Google jusqu'à 31B paramètres
Qwen3.6-Plus : programmation agentique et multimodalité
Qwen3.5-Omni : l'IA génère du code à partir de vidéo
Gemini 3.1 Flash Live pour les agents vocaux
TurboQuant : cache KV 3 bits pour LLM sans pertes
DRAGOn : test des systèmes RAG sur données dynamiques
Grands Modèles de Langage : Bases et Pratique
Ingénierie des prompts pour LLM : Techniques et Structure
Exécution de MoE GPT-OSS-120B sur GPU 6 GB jusqu'à 30 t/s
Compression de GLM-5.1 sur 16 GB VRAM : astuces GQA
La diversité des erreurs l'emporte sur la qualité dans les ensembles ML
DiffQuant : optimisation Sharpe dans un simulateur différentiable
Self-attention et multi-head dans les transformers
Augmentation Bbox dans Albumentations : formats et erreurs
Induction Heads sur TinyStories : formation faible
Verrou de Confirmation dans les LLM-agents : test LOCK-R
Réseaux de Neurones et Multiplication : SwiGLU dans les Transformers
Physique des LLM-graphs : métriques F et rho
Calculs de tenseurs PHP : Accélération GPU